Does Data Preprocessing Affect Tree-Based Super Learners? An Investigation of Ensemble Optimization and Oracle Properties in Clinical Classification.
Questo studio dimostra che per gli ensemble Super Learner composti da algoritmi basati su alberi, il pre-processing dei dati produce miglioramenti trascurabili nelle prestazioni predittive e nel comportamento oracle nella maggior parte dei dataset clinici, suggerendo che tale pre-processing non sia universalmente necessario e debba essere guidato dalle caratteristiche specifiche del dataset.